圖/本報資料庫
科技生活

·a few seconds ago·責任編輯
#Google#Meta#AI 模型#Gemini#Muse Spark
圖/本報資料庫
圖/本報資料庫
商傳媒|責任編輯/綜合外電報導
摘要

Google 在本週稍早推出了兩款新的輕量級 AI 模型 Gemini 3.8 Flash 與 Gemini 3.8 Flash Cyber,主打提升推理、編程及資安防護能力。然而,Meta 也於同一天發表了其新模型 Muse Spark 1.3,並在獨立的 AI 性能評估中,以 62 分略勝 Google 的 59 分。

Google 於本週稍早發布了最新的輕量級人工智慧(AI)模型 Gemini 3.8 Flash 及其資安專用版本 Gemini 3.8 Flash Cyber。然而,就在同一天,Meta 也推出了其新款 AI 模型 Muse Spark 1.3,並在獨立的外部評測中,Meta 的新模型在 AI 性能評估指標上略勝 Google 一籌。

Google 表示,Gemini 3.8 Flash 是迄今發布的 Flash 系列模型中,智慧程度最高的旗艦模型。它在軟體工程、AI 代理任務及多步驟推理能力方面有所提升。Google 更宣稱,Gemini 3.8 Flash 在 DeepSWE v1.1 等特定編程評估中,表現超越了 OpenAI 的 GPT-5.6 Sol 和 Anthropic 的 Claude Opus 5 等大型模型,並在金融與法律分析任務中優於其他前沿模型。

Gemini 3.8 Flash Cyber 則專為網路安全任務設計,在偵測漏洞和自動修補方面展現強大能力。Google 指出,它在 Chrome 瀏覽器漏洞修補測試中,產生的修補程式碼準確度比現有最佳商用模型高出 2.6 倍,並能於兩小時內完成 Google Cloud 先前需數月才能完成的漏洞偵測任務。Google 的 Gemini 3.8 Flash 定價與先前模型相同,推廣費率為每百萬輸入 Token(模型處理的最小資訊單位)0.75 美元,每百萬輸出 Token 3.75 美元。

值得注意的是,Google 近期不斷縮短輕量級模型的發布週期,包括 7 月 21 日的 Gemini 3.6 Flash 與上月 13 日的 Gemini 3.7 Flash。這次發布距離 Google 上一次推出 Flash 系列模型僅隔三週,顯示 Google 正積極加快輕量級 AI 模型的更新速度。然而,其高效能模型產品線的發展卻顯得停滯。原定於今年 6 月發布的下一代旗艦模型 Gemini 3.5 Pro 仍處於合作夥伴測試階段,而上一個 Pro 系列模型 Gemini 3.1 Pro 則是在今年 2 月發布。部分觀察家推測,Google 可能會跳過 3.5 Pro,直接推出 Gemini 4.0 Pro。

在 AI 模型性能評估方面,Google 的 Gemini 3.8 Flash 在外部獨立評估中獲得 59 分。同日發布的 Meta Muse Spark 1.3 則在 Artificial Analysis Intelligence Index(AAII,AI 模型性能評估指標)中拿下 62 分,與 Anthropic 的 Claude Fable 5.1 高性能配置並列第三,比 Gemini 3.8 Flash 高出 3 分。Meta 指出,Muse Spark 1.3 在編程與多工具代理能力方面均有所提升,其工具調用次數減少約 20%,Token 使用量也減少約 25%。